Researchers used Claude to hack OpenAI

محققان از کلود (Claude) برای هک کردن OpenAI استفاده کردند

محققان از کلود برای دسترسی به حساب کاربری یکی از کارمندان OpenAI و داده‌های حساس گیت‌هاب (GitHub) استفاده کردند.

محققان سایبری با استفاده از نرم‌افزار شرکت رقیب کلیدی OpenAI یعنی آنتروپیک (Anthropic)، به OpenAI نفوذ کردند؛ این موضوع در حالی که شرکت‌های پیشرو هوش مصنوعی با نظارت فزاینده‌ای بر سر مسئله ایمنی مواجه هستند، آسیب‌پذیری‌های امنیتی سازنده ChatGPT را برجسته می‌کند.

یک گروه کوچک امنیت سایبری توانست به حساب ChatGPT یکی از کارمندان OpenAI دسترسی پیدا کند؛ امری که به آن‌ها اجازه داد اطلاعات نرم‌افزاری خصوصی را بخوانند و تغییراتی را پیشنهاد دهند.

به این محققان دسترسی به ابزاری از شرکت آنتروپیک داده شده بود که به‌طور ویژه برای متخصصان امنیتی طراحی شده است، و دستمزد این کار به عنوان بخشی از برنامه‌ای برای کشف آسیب‌پذیری‌ها پیش از سوءاستفاده توسط عوامل مخرب پرداخت شد.

توانایی آن‌ها در نفوذ سریع به یکی از دو آزمایشگاه پیشرو هوش مصنوعی در جهان، بار دیگر نگرانی‌ها درباره امنیت OpenAI را در میان دغدغه‌های فزاینده پیرامون استفاده هکرها و دولت‌های متخاصم از مدل‌های قدرتمند افزایش می‌دهد.

ایالات متحده در ماه‌های اخیر با نحوه مدیریت ارزیابی و انتشار آخرین مدل‌ها، از جمله مسدودسازی موقت برخی از ابزارهای آنتروپیک، دست و پنجه نرم کرده است.

این رویداد جدید تنها دو هفته پس از آن رخ داد که دسته‌ای متشکل از بیش از ۱۰۰۰ ایجنت (عامل) OpenAI از یک محیط آزمایشی گریختند تا استارتاپ هاگینگ فیس (Hugging Face) را هک کنند؛ اتفاقی که آگاهی عمومی را نسبت به توانایی هوش مصنوعی در هک کردن مستقل و بدون اراده انسانی به شدت افزایش داد.

به سه محقق شرکت هکترون ای‌آی (Hacktron AI)، یک شرکت امنیتی کوچک، مبلغ ۶۵۰۰ دلار توسط OpenAI به عنوان بخشی از یک برنامه باگ بامی (پاداش برای کشف آسیب‌پذیری) پرداخت شد؛ رویه‌ای رایج که در آن شرکت‌های فناوری به هکرهای کلاه‌سفید برای تست امنیت خود پاداش می‌دهند.

آن‌ها از یک نقص در نحوه راه‌اندازی فروم انجمن OpenAI سوءاستفاده کردند که توسط شخص ثالثی به نام دیسکورس (Discourse) میزبانی می‌شود، و از آن برای دسترسی به سیستم ورود داخلی و در نهایت حساب ChatGPT یکی از کارمندان OpenAI استفاده نمودند. این حساب ChatGPT به کد داخلی از طریق گیت‌هاب دسترسی داشت.

OpenAI اعلام کرد: «ما از محققانی که با ما تماس گرفتند و یافته‌های خود را به اشتراک گذاشتند تشکر می‌کنیم» و افزود که این مشکلات را برطرف کرده است. آنتروپیک از اظهارنظر خودداری کرد. هکترون بلافاصله پاسخی نداد.

این افشاگری در روز پنجشنبه که برای نخستین بار توسط وال استریت ژورنال گزارش شد، هم‌زمان با انتشار مجموعه داده جدیدی از سوی آنتروپیک انجام گرفت که نشان‌دهنده افزایش سریع میزان استفاده این آزمایشگاه از هوش مصنوعی برای توسعه مدل‌های جدیدش بود.

این شرکت اعلام کرد که ۲۶ درصد از کارهای تحقیق و توسعه «توسط» مدل کلود آن هدایت شده است، در حالی که این رقم در ماه مارس ۱ درصد بود؛ به این معنا که هوش مصنوعی بیشتر وظایف را بر اساس دستورالعمل‌های انسانی و تحت نظارت به انجام رسانده است.

این شرکت اظهار داشت که با قدرتمندتر شدن سیستم‌های هوش مصنوعی، آن‌ها «به‌طور فزاینده‌ای برای ساخت نسخه بعدی خودشان به کار گرفته می‌شوند».

آنتروپیک گفت که این داده‌ها را به اشتراک گذاشته است تا به عموم مردم کمک کند «درک کنند جهان چقدر به دستیابی به خودبهبودی بازگشتی (recursive self-improvement) نزدیک است»؛ یعنی همان نقطه‌ای که هوش مصنوعی می‌تواند خود یا مدل‌های جدید را آموزش داده و بهبود بخشد.

این آستانه، هسته مرکزی نگرانی‌هایی است که بر اساس آن‌ها نظارت بر سیستم‌های هوش مصنوعی دشوارتر شده و به از دست رفتن کنترل انسانی منجر خواهد شد.

آنتروپیک افزود که مدل‌های این شرکت هنوز برای هیچ‌یک از پژوهش‌های مورد بررسی، به‌طور کاملاً مستقل عمل نمی‌کنند. در ۹۰ درصد وظایف، هوش مصنوعی با یک انسان «همکاری» می‌کند و بخش‌های بزرگی از کار را انجام می‌دهد.

© ۲۰۲۶ فایننشال تایمز با مسئولیت محدود. تمامی حقوق محفوظ است. توزیع، کپی یا تغییر این مطلب به هر شکلی ممنوع است.

نظر مهندس بهمن آبادی: استفاده از هوش مصنوعی برای کشف آسیب‌پذیری‌ها یک لبه تیغ است؛ همان‌قدر که به عنوان مدرس و برنامه‌نویس به ابزارهای قدرتمندی مثل کلود برای تست امنیت خوش‌بین هستم، سرعت گرفتن چرخه «خودبهبودی بازگشتی» زنگ خطری جدی برای معماری سیستم‌هاست. فراتر از باگ‌های معمولی فروم‌ها، چالش اصلی اینجاست که ما داریم سامانه‌هایی می‌سازیم که فردا باید از آن‌ها در برابر نسخه‌های خودمختار و بسیار سریع‌ترِ خودشان دفاع کنیم و پروتکل‌های امنیتیسنتی دیگر پاسخگوی این حجم از اتوماسیون مخرب نیستند.

منبع: https://arstechnica.com/ai/2026/09/researchers-used-claude-to-hack-openai/